Kimi 新模型 K2.8 Preview 全量上线!综合性能逼近 K3!
Kimi 新模型 K2.8 Preview 全量上线!综合性能逼近 K3!Kimi K2.8 Preview 编程模型全量上线 Kimi Code,支持 1M 超长上下文并向所有会员档位开放,综合性能接近 K3,默认采用 Max 思考档位,编码和智能体能力较 K2.7 Code 有所提升。
搜索
Kimi K2.8 Preview 编程模型全量上线 Kimi Code,支持 1M 超长上下文并向所有会员档位开放,综合性能接近 K3,默认采用 Max 思考档位,编码和智能体能力较 K2.7 Code 有所提升。
之前「elsewhere」写过 Kimi 的C轮融资,那笔由 IDG 领投的交易,堪称VC在黎明前的惊鸿一注。但回顾 Kimi 的融资故事,真正将杨植麟送上大模型牌桌的,是更早、也更大的一笔来自阿里的钱。
与虎嗅对谈当天,他正以 3000 万美元估值推进第二轮融资,腾讯、阿里、美团等多家大厂战投均已接触。这位 94 年的创业者是南方科技大学 2019 届毕业生,先后在微信、TikTok 负责搜索推荐业务,2025 年 5 月辞任 Kimi AI 搜索负责人,放弃千万期权下场 All in AI 婚恋。
一块 8.24GB 内存的 CPU,一个 2.78 万亿参数的大模型,甚至不需要显卡,Kimi K3 就这么水灵灵地跑起来了。
最近,Wafer AI 在 AMD MI355X 上部署了 Kimi K3。结果是,原本需要 16 张 NVIDIA B200、横跨两台服务器运行的模型,在一台配备 8 张 MI355X 的 AMD 服务器中就能完成部署。
有人总结,运行 Kimi K3 其实很容易,只需要 1.5TB GPU 内存、大约 8 张 H100,以及一座小型变电站。一名开发者拿出一台 128GB 统一内存的 M5 Max,直接加载 Kimi K3 发布在 Hugging Face 上的官方 MXFP4 权重。
最近有个挺有意思的对比实验,来自 Composio 团队。他们用同一个模型 Kimi K3,分别放进三个不同的 agent 框架(harness)里跑 ——Claude Code、Hermes 和 Kimi Code—— 一共测了 28 个完全相同的任务。
起底 K3 背后核心极客天团,人均扛起 7 亿估值!
“推理轻量化,训练提效 25%,前端效果同样惊艳。 ”
最近,月之暗面 kimi 正式开源 Kimi K3 完整模型权重,Kimi K3 是一款总参数量达 2.8 万亿、上下文窗口达 100 万 token 的 MoE 大模型,更是全球首个落地的近 3 万亿参数级开源大模型,引起业界热议。